如果你真的一路看到 Day 30,希望你現在得到的不是一張更長的 Agent 技術清單。 你開始有能力在面對一個新的 Agent 問題時,先問:「它到底失敗在哪...
前面 28 天,我們一路把 Agent Harness 拆成約 20 種機制。 到這裡,很容易進入一種「架構焦慮」。 Agent 表現不好時,第一個反應常常是:...
Day 25 到 Day 27,我們看了三種很不一樣的 Agent Harness。 Claude Code: 完整 Production Coding Ha...
前兩天我們看了兩個很完整的系統。 Day 25 的 Claude Code 告訴我們: 一個 Model 要安全地修改真實 Repository,需要完整的...
Day 25 我們看 Claude Code。 它最適合研究: 一個 Production Coding Agent 如何安全地在真實 Repository...
前 24 天,我們把 Agent Harness 拆成很多獨立機制。 從 Day 25 開始,我們不再新增新的抽象層。 接下來要做的是反過來看真實 Agent:...
DeepSeek 在 2026 年 8 月 13 日開源 DeepSeek Harness。到 8 月 24 日,GitHub 已經累積約 19.2 萬個 St...
前一天我們談 Loop Engineering。 核心是把: Agent Loop Verification Loop Event Loop Improveme...
前一天我們談 Evaluation。 到這裡,我們已經能回答: 這次修改,真的讓 Agent 變好了嗎? 但很多 Agent 系統仍然有一個隱藏問題。 Ag...
前一天我們談 Observability。 Observability 可以回答: Agent 做了什麼 呼叫哪些 Tool 哪裡失敗 花多少 Token 花...
前面 20 天,我們已經把一個 Agent 從最小 Loop 一路擴展到: Tool Runtime Permission / Approval / Sand...
前一天我們談 Autonomy。 當 Agent 已經能長時間自主執行,下一個最常見需求就是: 接更多外部能力。 例如: GitHub Slack Gma...
前一天我們談 Agent Protocol。 現在 Agent 已經可以: 接 Task Background 執行 Schedule Spawn Subag...
前一天我們談 Multi-Agent Coordination。 當多個 Agent 開始互相傳遞結果時,下一個問題是: 它們要用什麼格式溝通? 最簡單的做...
前一天我們談 Worktree Isolation。 現在每個 Agent 已經可以有: 自己的 Task 自己的 Context 自己的 Permissio...
前一天我們談 Scheduling。 當 Agent 可以 Background、Recurring、Parallel 執行後,Coding Agent 很快會...
前一天我們談 Background Execution。 有了 Queue、Worker、Task State 之後,Agent 已經可以在使用者離線後繼續執行...
前一天我們把 Agent Task 變成一個真正有 State 的系統。 下一個問題自然是: 如果任務要跑 20 分鐘,誰來執行? 很多 Demo 會直接在...
前一天我們談 Error Recovery。 當 Agent 開始有 Retry、Fallback、Approval、Replan、Human Handoff...
前一天我們談 System Prompt Assembly。 核心觀念是: System Prompt 不是一份固定文件,而是 Harness 根據目前狀態動...
前一天我們談 Memory。 Memory 的核心不是把所有歷史永久保存,而是決定: 什麼值得記 要記成什麼 什麼時候 Recall 什麼時候更新、合併或忘掉...
前一天我們談 Context Management。 核心觀念是: Storage 負責不遺失資料,Context 負責讓模型看見現在最重要的資料。 但這還...
前一天我們談 Skills 與 Progressive Disclosure。 核心觀念是: Context 是工作區,不是倉庫。 Agent 不需要一開始...
前一天我們談 Subagent。 Subagent 的價值,不是單純增加 Agent 數量,而是建立更乾淨的 Context、責任、權限與結果邊界。 今天要處理...
前一天我們談 Planning。 Planning 的核心不是列出漂亮步驟,而是把任務轉換成可以追蹤、驗證、重新規劃的執行狀態。 當 Plan 變得更大時,下一...
AI Agent 可能是近年最容易出現新工程名詞的領域。 我們才剛學會 Prompt Engineering,接著又出現: Context Engineeri...
很多團隊評估 Agent 的方法,其實還停留在評估 Chatbot。 準備一組問題、跑一次模型、比較輸出,再算出一個正確率。 但 Agent 處理的通常不是單...
前幾天我們逐步建立了一個最小 Agent 架構。 目前系統已經有: Agent Loop Tool Runtime Schema Validation Per...
前幾天我們逐步建立了 Agent 的基本控制平面: Agent Loop Tool Runtime Permission Approval Sandbox H...
前一天我們拆解了 Tool Calling 和 Tool Runtime。 模型產生 Tool Call,只代表它提出一個行動請求。 真正的 Tool Runt...
iThome鐵人賽